Type: entity
Confidence: 0.70
Created: 2026-04-20
Updated: 2026-04-20
Tags: persondeep-learningreinforcement-learning强化学习

Volodymyr Mnih

概述

深度学习与强化学习研究者,DQN(深度 Q 网络)的主要发明者,开创了深度强化学习领域。

关键内容

  1. DQN 论文(2013):发表《Playing Atari with Deep Reinforcement Learning》,首次将 卷积神经网络(CNN) 与 Q-learning 结合,使 AI 能够从像素输入直接学习玩 Atari 游戏。
  2. 经验回放:引入经验回放机制,打破数据相关性,稳定深度强化学习训练,这一技术成为后续 PPO算法的基础。
  3. 历史影响:DQN 证明了深度学习可以与强化学习结合,直接促成了 AlphaGo 等后续突破。

来源

相关